AFS AI Hub 雲端版模型清單
| 模型名稱 | 短簡介(10字內) | 發行者 | 檔案大小 | 模型類別 | 模型格式 / 精度 | 模型參數量 | 上下文長度 |
|---|---|---|---|---|---|---|---|
| Llama3.3-FFM-70B | 繁中強化的語言模型 | TWAI | 131.43GB | 語言模型 | FP16 | 70B | 32K |
| Llama3.2-FFM-11B | 繁中強化的多模態模型 | TWAI | 19.89GB | 視覺語言模型 | FP16 | 11B | 32K |
| Llama3.1-FFM-8B | 繁中強化的語言模型 | TWAI | 14.97GB | 語言模型 | FP16 | 8B | 32K |
| FFM-Embedding-v2.1 | 繁中強化的向量模型 | TWAI | 2.32GB | 向量模型 | FP16 | 1B | 8K |
| gpt-oss-20B | OpenAI推理模型 | OpenAI | 38.46GB | 推理模型 | MXFP4 | 20B | 128K |
| gpt-oss-120B | OpenAI推理模型 | OpenAI | 182.32GB | 推理模型 | MXFP4 | 120B | 128K |
| llama-nemotron-rerank-vl-1b-v2 | 精準文本再排篩選模型 | NVIDIA | 3.14GB | 再排序模型 | BF16 | 1B | 8K |
| llama-nemotron-embed-vl-1b-v2 | 高效輕量文本向量模型 | NVIDIA | 3.14GB | 向量模型 | BF16 | 1B | 10K |
| llama-embed-nemotron-8b | 高精度大型文本向量模型 | NVIDIA | 14GB | 向量模型 | BF16 | 7.5B | 32K |
| gemma-4-31B-it | 高效能稠密型多模態模型(尚未啟用影片推理) | 58.28GB | 多模態模型 | BF16 | 31B | 256K | |
| gemma-4-26B-A4B-it | 高效能多模態混合專家模型(尚未啟用影片推理) | 48.1GB | 多模態模型 | BF16 | 26B | 256K |